登入
關鍵字
#AI 能力
官方認證
RexAA
2026/09/18
•
那個教 ChatGPT 說話的人,做了一個「啞巴」模型
嘴閉上了,腿腳快得飛起! AI 圈子裡最懂怎麼讓模型「開口聊天」的人,現在決定剝奪大模型的語言能力。 這位前 OpenAI 研究員、ChatGPT 的共同發明者 Diogo Almeida,在潛行兩年後帶著他的新公司 TypeSafe AI 和 4000 萬美元融資回到牌桌。他們發佈的全新模型 Jev,既不能寫打工人的周報,也不能陪使用者深夜長聊。它甚至連一個標點符號都吐不出來。 TypeSafe 創始人 Diogo Almeida|圖片來源:X
科技
#AI模型
#AI Agent
#ChatGPT
讚
留言
分享
官方認證
RexAA
2026/09/14
•
Anthropic CEO Dario Amodei 最新長文全文:AI 發展太快,必須讓其定速發展!
Dario Amodei 的核心不是反對 AI,而是主張:在遞迴自我改進加速和 Agent 風險顯現後,以可核驗的駐場評估為起點,先在民主國家內部協調,再爭取全球協調,給前沿能力推進定速,讓對齊和治理跟得上;同時以保持美國領先為前提。定速不是暫停,而是把多出來的時間用於安全、對齊、可解釋性和評估,確保 AI 的好處以正確方式兌現。 核心內容 一、核心命題:必須給前沿 AI“定速” Dario Amodei 的核心主張是:必須放慢提升 AI 模型能力的速度,即“給前沿定速”。
科技
#Anthropic CEO
#Dario Amodei
#AI 模型能力
讚
留言
分享
官方認證
北風窗
2026/08/03
•
突發!DeepSeek-V4-Flash 正式發佈並開源核心技術深度洞察!
2026年8月2日,深度求索公司正式宣佈其旗艦大模型DeepSeek-V4-Flash的穩定版本全面上線並同步開源。 這一事件不僅標誌著中國AI公司在大模型領域的重大技術突破,更以其極致的效率、顛覆性的成本結構和強大的Agent能力,為全球AI產業的發展路徑投下了一枚深水炸彈。 本文將深入剖析這一模型背後的核心技術革新,解讀其在多維度Agent任務中的卓越表現,並從產業鏈視角審視其可能引發的深遠影響。 一、 技術架構:輕量MoE與注意力機制的革命性融合
科技
#DeepSeek-V4-Flash
#MoE
#Agent能力
讚
留言
分享
官方認證
RexAA
2026/07/30
•
《AI產業全景圖譜》新書節選|基準之戰:測試體系與模型話語權的角逐
轉自中信智庫、中信建投證券研究發展部出品 武超則等著《AI產業全景圖譜:技術範式、投資機遇與未來生態》,中信出版集團。 《AI產業全景圖譜》新書第一章“模型為王:AI 新範式的確立與演進”內容節選——基準之戰:測試體系與模型話語權的角逐。 基準測試為整個大模型行業提供了一個標準化的目標和一把統一的“標尺”。通過科學適當的基準測試手段,能夠客觀量化地衡量大模型的性能,精準地定位下一階段研發迭代的重點方向,有力地約束大模型安全可控。不同於傳統的自然語言處理模型,大模型具有複雜性、多樣性、開放性,同時還具備一定的泛化特徵。因此在大模型充分發展之前,此前用於自然語言處理工具的測試手段並不適用,需要建構全新的基準測試框架,而這種測試框架也將隨著大模型自身能力的不斷升級而持續迭代。 根據各類測試結果,很多公開的排行榜(如Hugging Face的Open LLM Leaderboard和LMSys的Chatbot Arena)將基準測試的驅動作用進一步放大,激勵著全球開發者和公司不斷最佳化模型。隨著模型規模的擴大,模型會表現出一些在小模型上不存在的“湧現能力”,如思維鏈推理。基準測試是系統性發現、追蹤和研究這些能力的關鍵工具。基準測試能幫助我們揭示和量化模型的潛在風險,如偏見、毒性內容生成和對特定攻擊的脆弱性。
科技
#AI產業
#大模型
#推理能力
讚
留言
分享
官方認證
北風窗
2026/04/19
•
國內首顆!完成流片!
北海永星電子有限公司(永星科技)是國家級高新技術企業,長期深耕於航天、航空、通訊等高端領域。公司以解決高端晶片“卡脖子”問題為己任,其投資建設的銀河晶片產業園,致力於成為國內領先的宇航級晶片與高端元器件研發製造基地,產品已廣泛應用於多項國家重大工程及商業航天項目,是推動中國商業航天產業自主創新發展的重要力量。國內首顆!永星科技高性能宇航級抗輻照晶片流片成功,破局商業航天“芯”瓶頸!北京,2026年4月18日 —— 國內商業航天關鍵核心器件迎來重大突破。北海永星電子有限公司(以下簡稱“永星科技”)今日正式宣佈,其研發的高性能宇航級抗輻照數字訊號處理器(DSP)已成功完成流片。這是國內首顆將高速衛星通訊基帶處理與星上人工智慧(AI)計算能力整合於一體的抗輻照系統級晶片(SoC),旨在解決中國大規模低軌衛星星座建設中對高算力、低功耗、高可靠性的迫切需求,為中國商業航天提供了低成本、高可靠的國產“芯”選擇。 (芯榜)
科技
#永星科技
#DSP
#AI計算能力
讚
留言
分享
官方認證
RexAA
2026/04/06
•
黃仁勳最新訪談:要想成事,這4點遠比智力更重要!
AI 浪潮之下,工作方式、組織形態與個人價值正迎來根本性重構。在最近的一次深度訪談裡,一手推動全球 AI 革命的黃仁勳,說了一句顛覆所有人認知的話:智能正在成為一種廉價的商品。在 AI 時代,人類真正的核心競爭力,從來都不是智商,而是人性。這位全球任期最長的科技公司CEO,手下管著60位各領域頂尖的專家,每一個人在自己的專業賽道上,智商和能力都遠超他本人。但黃仁勳這位掌舵人,帶著輝達從一家瀕臨破產的顯示卡公司,長成了如今市值4萬多億美元的 AI 時代第一大廠。這篇文章,我們就從黃仁勳的親身經歷和底層思考裡,拆透 AI 時代最本質的生存法則:當智能變成一種廉價商品,到底什麼才是一個人、一家企業,真正不可替代的護城河。一、你拚命內卷的“智商”,正在被AI變成廉價商品以前我們覺得,能寫一手好程式碼的程式設計師、能精準分析財報的金融分析師、能快速出全案的品牌策劃,都是靠高智商吃飯的 “不可替代者”。但現在,AI能在幾分鐘內完成這些工作,成本不到人工的百分之一,精準率甚至更高。黃仁勳說,我們一直把“智能”這個詞過度浪漫化了,從本質上看,它就是感知—理解—推理—計畫的閉環,是一套功能性的動作。AI正在做的,就是把這套功能性的智力動作,徹底工業化、標準化、廉價化。你拚命內卷的知識儲備、計算能力、邏輯推理,只要是能被拆解成流程、被標準化的,AI都能比你做得更快、更好、更便宜。很多人焦慮AI會替代自己,其實換個角度想,是把自己繫結在了AI最擅長的標準化智力勞動上。你和AI比算力、比記憶力、比標準化的邏輯推理,就像當年手工紡織工人和蒸汽機卷產量一樣,從一開始就輸了。就像工業革命把手工勞動者從標準化的體力勞動裡解放出來,AI革命,正在把我們從標準化的智力勞動裡解放出來。既然標準化的智商已經成了廉價商品,那在AI時代,我們真正要拼的,到底是什麼?二、黃仁勳用34年驗證出,AI永遠替代不了的4種核心能力1. 遺忘痛苦的能力,以及相信未來的韌性所有瞭解輝達歷史的人,都知道CUDA平台,但很少有人知道,當年為了做CUDA,輝達差點破產。在CUDA誕生之前,輝達只是一家做遊戲顯示卡的公司,靠著GeForce系列產品站穩了腳跟。但黃仁勳從一開始就知道,只做單一功能的產品,路只會越走越窄。他想做的是通用的加速計算平台,CUDA就是這個夢想的核心。但這個決策,在當時幾乎是“自殺式”的。把CUDA放進每一塊GeForce顯示卡裡,會極大增加晶片成本,直接吞掉公司全部的毛利。當時輝達的市值大約在70億美元,而CUDA推出後,市值一路跌到了15億美元,全公司上下和資本市場,全是質疑的聲音。換做任何一個人,面對這樣的局面大機率都會止損放棄。但黃仁勳扛住了所有壓力,硬生生把這個決策堅持了十幾年,最終讓CUDA成了AI時代全球計算的核心底座,也讓輝達完成了從顯示卡公司到AI基礎設施巨頭的躍遷。很多人問他,到底是怎麼扛過那段至暗時刻的?他在訪談裡說了一句很有意思的話:AI學習最重要的屬性,就是系統性遺忘。人也是一樣,真正的韌性,從來不是扛住痛苦的能力,而是快速遺忘痛苦的能力。面對挫折和焦慮,他永遠只做三件事:第一,把問題徹底拆解,分開那些是可控的、那些是不可控的;第二,快速遺忘那些不可控的失敗、尷尬、羞辱,不把它們背在身上;第三,把所有精力,放到一件現在就能做的、可控的小事上,立刻行動。你看,AI能做最精準的機率計算,能做完美的邏輯推演,但它永遠不會有 “明知大機率失敗,依然願意賭上整個公司堅持” 的勇氣,不會有摔得粉身碎骨,依然能爬起來繼續走的堅定與韌性。AI時代,不確定性只會越來越多,比起完美的規劃,能扛事、能遺忘、能重新出發的韌性,才是你最基本的生存底氣。2. 共情與信任的能力這次訪談裡,黃仁勳講了一句輕描淡寫,但是讓商業圈大受震撼的話:輝達和台積電合作了30年,涉及數百億美元的生意,但雙方之間沒有一份正式的合同。不止是台積電,黃仁勳能提前3年說服全球頭部記憶體廠商,在HBM記憶體(筆記俠註:一種先進的半導體儲存技術,主要用於滿足高性能計算、人工智慧、圖形處理等領域對記憶體頻寬和傳輸速度的極高需求)還只用於小眾超級電腦、幾乎沒有商用場景的時候,就砸下數十億美元擴產。很多人覺得,這是因為輝達的行業地位,是因為利益繫結。但黃仁勳自己說,這靠的不是合同約束,不是利益算計,而是基於共同願景的信任。黃仁勳做所有事,都是把自己的戰略、對未來的判斷,毫無保留地分享給合作夥伴,從第一性原理出發,給他們講清楚 “為什麼要做這件事”,給他們充分質疑的機會,給他們足夠的尊重。黃仁勳會告訴他們,未來3年行業會發生什麼,這個投資會給他們帶來什麼長期價值。對內管理也是一樣。他管著60個直屬下屬,全是各領域的頂尖專家,但他從來不開一對一會議,所有問題都放在公開會議上,所有人一起推演、一起解決。有人問他,這麼多人,一對一溝通根本忙不過來,不怕資訊不對稱嗎?他說:恰恰是一對一會議,才會造成資訊不對稱。所有問題放在檯面上,所有人都能聽到上下游的訴求,都能理解彼此的難處,都能一起參與決策,這才是最高效的協作。而這一切的前提,就是信任。AI能把利益帳算到極致,能做最精準的博弈分析,能寫出滴水不漏的完美合同,雖然AI能把一件件事情做好,但人與人之間必須建立在信任的基礎上才能把一件件看似難以聯絡在一起的事情打通,它永遠理解不了“信任”兩個字的重量。商業的本質,是人和人的協作。一份合同,只能約束對方不做壞事,只能守住合作的底線;但一份信任,能驅動一群人,一起做成一件沒人做過的大事,能拉高合作的上限。AI時代,資訊越來越透明,計算越來越容易,但真正稀缺的,永遠是別人願意毫無保留地和你背靠背的信任。注意,AI有做事的能力,但是AI不是生命,無法理解生命之間不只是理性才能協同。3. 願景與意義感黃仁勳在訪談裡說,他的60個直屬下屬,個個都是各自領域的超人,每一個人在專業上,都比他聰明得多。很多人都好奇,一個專業能力不如所有下屬的人,憑什麼能帶著這家公司,做成兆級的事業?答案很簡單:他能給所有人一個共同的願景,能定義 “我們為什麼要做這件事”,能給所有的技術、所有的算力,找到一個真正有意義的方向。他在訪談裡說,未來全球能程式設計的人,會從現在的3000萬,暴增到10億。因為程式設計的本質,早就不是寫一行行程式碼了,而是給電腦提需求、定規格、描述你想要實現的目標。這件事,AI能幫你完成99%。但AI永遠不能定義的,是“我們為什麼要寫這個程式碼”、“我們要解決什麼人的什麼痛點”、“我們要給世界帶來什麼改變”。輝達能從一家遊戲顯示卡公司,進化成AI時代的全球頂尖公司,靠的不是黃仁勳比別人更懂晶片設計,而是他從一開始,就看準了“加速計算”這個方向,想給全世界的創新者,提供最強大的算力基礎設施。那怕在最艱難的時候,這個願景也從來沒變過。AI永遠不會有“我想改變世界”的願望,永遠不會有“我想幫使用者解決一個痛點”的初心,永遠不會有“我想給社會創造價值”的意義感。而所有偉大的企業、偉大的產品,本質上都是被願景和意義感驅動的。AI是一個無限強大的工具,但工具永遠需要人來定義方向。沒有方向的算力,再強也毫無意義;沒有意義的智能,再先進也走不遠。AI時代,最不缺的就是能幹活的工具,最稀缺的永遠是能定義方向、賦予意義的人。4. 謙遜與成長力那怕現在成了全球頂級的CEO,黃仁勳在訪談裡,依然坦然說起自己的第一份工作是在餐廳刷廁所。他從來沒有“成功者的傲慢”,永遠保持著初學者的心態,永遠在向所有人學習。最能體現這一點的,是他對“繼任計畫”的理解。很多人都知道,黃仁勳以“不相信繼任計畫”聞名。有人說,這是因為他貪戀權力,覺得自己能一直幹下去。但他在訪談裡,給出了完全不一樣的答案:“我不相信繼任計畫,不是因為我是永生的。而是因為如果你真的關心公司在你之後的未來,你今天最該做的事,不是找一個接班人,而是持續地、毫無保留地傳遞知識、資訊、洞察力、技能和經驗,賦能你身邊的每一個人。”他的每一次會議,都是一次公開的推理會議。他不會直接下達指令,而是會把自己的思考邏輯、判斷依據、甚至是顧慮和不確定性,全部攤開給團隊看,帶著所有人一起推演,一起最佳化,一起成長。他學到的任何東西,從來不會在自己的腦子裡停留超過一秒鐘,立刻就會分享給團隊。他討厭“持續改進”的思維,因為這種思維本質上是默認了“現在的做法是對的”,只能小修小補。而他永遠會回到零,回到第一性原理,問自己:這件事為什麼要這麼做?如果從頭開始,以今天的技術和條件,我們能做成什麼樣?這種思維的前提,就是永遠保持謙遜,永遠不被自己過去的經驗和優越感困住。所以,真正的長期主義,本質上就是持續成長的能力,就是永遠能打破自己、重構自己的能力。AI時代,知識更新的速度只會越來越快,比起你已經掌握的知識,永遠保持謙遜、永遠能成長的能力,才是決定你能走多遠的核心。三、AI時代,修煉 “人性競爭力” 的4句話1. 把工作分成兩類:一類是標準化智力任務:比如做資料統計、寫常規程式碼、整理資料、套範本做方案、重複的報表分析;另一類是人性價值任務:比如和使用者聊真實的需求痛點、和團隊做深度溝通、制定業務的長期方向、解決非標準化的複雜問題、給客戶提供有溫度的服務。未來,要把你80%的精力,放到後者上面。AI能幫你高效完成前者,但後者才是你不可替代的核心價值。2. 比起完美的規劃,能讓你在不確定性裡站穩腳跟的,永遠是立刻行動的韌性。3. 不管是對合作夥伴、團隊同事,還是你的客戶,放棄零和博弈和 “算計到底” 的小聰明。和客戶合作,多做一件超出預期的事,那怕只是多給一個實用的小建議;和同事協作,多一分坦誠的溝通,少一點背後的算計;和夥伴相處,多站在對方的角度考慮問題,守住自己的底線,也給對方足夠的尊重。4. 永遠保持 “初學者心態”,放棄你的智商優越感。結語今天我們深嵌於一個新的時代,科技、經濟、哲學、政治都在經歷持續變革和深刻重塑的複雜社會與商業環境之中,而真正困住絕大多數人的核心挑戰,恰恰是:我們的認知框架、組織形態和行動邏輯,還停留在“前全球化時代”、“前AI時代”。 (筆記俠)
科技
#AI
#黃仁勳
#核心能力
讚
留言
分享
官方認證
RexAA
2026/02/25
•
Gemini 3.1 Pro突襲:推理能力翻倍,Google打響AI"小步快跑"第一槍
引言當行業還在期待GPT-5.3時,Google用一場".1"版本號革命重新定義了AI迭代節奏。2026年2月24日凌晨,Google突然發佈Gemini 3.1 Pro大模型,這是其首次採用".1"小版本號,但升級幅度卻遠超預期。在ARC-AGI-2基準測試中,Gemini 3.1 Pro得分77.1%,是Gemini 3 Pro(31.1%)的2倍還多。這一突破不僅刷新了Google自身的技術紀錄,更標誌著大模型行業正式進入"高頻小步快跑"的新時代。更關鍵的是定價策略:每百萬token輸入僅2美元,輸出10美元,這一價格直接對標Anthropic Sonnet 4.6,在保持性能領先的同時實現了成本的大幅最佳化。Google用行動證明,AI競爭不再是"參數軍備競賽",而是"效率與速度的比拚"。01 技術突破:推理能力的量子躍遷Gemini 3.1 Pro最引人注目的突破在於推理能力的翻倍提升。傳統大模型升級往往聚焦於參數規模或多模態能力,而Google此次選擇了更艱難的路徑——從根本上提升模型的邏輯推理和問題解決能力。ARC-AGI-2基準測試的77.1%得分意味著什麼?這一測試專門評估AI系統的抽象推理能力,要求模型從有限示例中歸納出通用規則,並應用於全新場景。77.1%的得分不僅超越了所有前代Gemini模型,更接近了人類專家的表現水平。對比之下,GPT-5.2在同一測試中的得分為68.3%,Claude Opus 4.6為72.8%。多模態能力的全面進化同樣令人印象深刻。Gemini 3.1 Pro支援100萬token超長上下文窗口,能夠一次性處理整本書等級的文件或大型程式碼庫。在創意程式設計方面,模型能夠直接生成3D版"椋鳥群飛"動畫,並支援手勢追蹤互動,實現了從靜態內容生成到動態互動體驗的跨越。vibe coding能力的同步增強為開發者帶來了全新體驗。模型能夠更好地理解程式碼背後的設計意圖和架構邏輯,而不僅僅是語法正確性。實測資料顯示,在處理複雜演算法重構、架構最佳化等任務時,Gemini 3.1 Pro的精準率比前代提升45%。02 行業意義:從"整數版本"到".1迭代"的範式轉變Google首次採用".1"小版本號,這一看似微小的變化背後,是AI行業發展邏輯的根本性轉變。高頻小步快跑成為新常態。傳統上,大模型迭代以整數版本為單位,升級周期長達數月甚至半年。Gemini 3.1 Pro的發佈預示著,未來AI能力的進化將更加頻繁、更加精細。預計未來6個月內,我們將看到更多".1"、".2"等級的快速迭代,而非傳統的整數版本更新。企業應用更新機製麵臨重構。對於依賴AI服務的企業而言,這意味著需要建立更敏捷的AI應用更新機制。傳統"一年一升級"的節奏將被打破,企業需要能夠快速適配模型能力的持續最佳化,保持競爭優勢。技術競爭維度更加多元。當版本迭代頻率提升,競爭不再侷限於"誰先發佈大版本",而是"誰能持續提供最優體驗"。這要求廠商在模型最佳化、工程效率、生態建設等多個維度保持領先。使用者受益程度顯著提升。更頻繁的迭代意味著使用者能夠更快享受到技術進步帶來的價值。無論是開發者工具的增強,還是消費級應用的體驗最佳化,都將以更快的節奏呈現給終端使用者。03 定價策略:性能領先下的成本最佳化Gemini 3.1 Pro的定價策略同樣體現了Google的戰略思考。每百萬token輸入2美元、輸出10美元的價格,在保持性能領先的同時,實現了對競品的成本優勢。對比分析顯示:相比Anthropic Sonnet 4.6(輸入3美元、輸出15美元),Gemini 3.1 Pro便宜33%相比OpenAI GPT-5.2 Turbo(輸入5美元、輸出15美元),成本優勢更加明顯在相同預算下,企業可以處理更多token量,實現更高的投入產出比中小企業市場成為重點。傳統高性能AI服務主要被大型企業壟斷,而Gemini 3.1 Pro的親民定價,意味著更多中小企業能夠負擔得起頂尖AI能力。這對於加速AI技術普惠、推動行業數位化轉型具有重要意義。開發者生態的吸引力增強。對於個人開發者和初創團隊而言,成本是選擇AI服務的關鍵考量。Gemini 3.1 Pro的性價比優勢,將吸引更多開發者加入Google生態,推動應用創新的繁榮。04 生態佈局:從模型到應用的全鏈路最佳化Gemini 3.1 Pro的發佈不是孤立事件,而是GoogleAI生態戰略的重要一環。Gemini App已全面上線。普通使用者可以通過Gemini App直接體驗新模型,享受比前代更精準的複雜問題解答能力。實測顯示,在處理數學證明、邏輯推理、專業諮詢等任務時,新模型的精準率和響應速度均有顯著提升。API服務的全面升級。開發者可以通過Gemini API快速接入新模型,享受推理能力翻倍帶來的效率提升。Google同時最佳化了API的穩定性和響應速度,確保企業級應用的高可用性。多模態創作工具鏈完善。結合Gemini 3.1 Pro強大的多模態能力,Google推出了全新的創意工具套件,支援"文生視訊+互動"的新型內容形式。這對於內容創作者、教育工作者、行銷人員等群體具有重要價值。企業級解決方案深化。針對金融、醫療、法律等垂直行業,Google提供了基於Gemini 3.1 Pro的定製化解決方案,幫助企業在保持資料安全的前提下,享受AI技術帶來的效率提升。05 競爭格局:三巨頭技術路線的分化Gemini 3.1 Pro的發佈,進一步凸顯了AI三巨頭技術路線的分化。Google的"推理優先"路線。通過持續最佳化模型的邏輯推理能力,Google正在建構差異化的技術優勢。在需要複雜問題解決、專業諮詢、科學計算等場景中,Gemini系列的表現日益突出。OpenAI的"通用能力"路線。GPT系列繼續強化其通用性和適應性,在保持各方面能力均衡的同時,通過規模效應降低成本。但整數版本迭代周期較長,可能面臨敏捷性挑戰。Anthropic的"安全與專業"路線。Claude系列在AI安全、專業任務處理上持續深耕,特別是在程式碼安全、法律合規等垂直領域建立了獨特優勢。但定價相對較高,可能限制其規模化應用。國產大模型的追趕壓力。雖然DeepSeek、智譜GLM-5等國產模型在特定領域表現出色,但在推理能力的系統性提升上仍需追趕。Gemini 3.1 Pro的發佈,為國產模型提供了重要的技術參考和競爭標竿。06 實測體驗:從"工具"到"思維夥伴"的進化對於一線使用者而言,Gemini 3.1 Pro帶來的體驗升級是實實在在的。複雜問題處理能力顯著提升。在測試中,模型能夠準確解答研究生等級的數學證明題,理解複雜的法律條文邏輯,提供專業的醫療諮詢建議。這種能力的提升,讓AI從簡單的資訊檢索工具,進化為真正的"思維夥伴"。長文件理解更加精準。得益於100萬token的上下文窗口,模型能夠準確理解整本書、大型程式碼庫、複雜研究報告的內容。在處理學術論文審稿、程式碼架構評審等任務時,表現接近人類專家水平。創意表達更加豐富。在內容創作測試中,模型不僅能夠生成高品質的文字內容,還能夠創作互動式動畫、設計複雜的資料可視化圖表、製作專業的簡報。這種多模態創作能力,為創意工作者提供了全新的工具。響應速度持續最佳化。官方資料顯示,Gemini 3.1 Pro的響應時間相比前代縮短30%,在處理複雜推理任務時,使用者能夠感受到明顯的流暢度提升。也看到了Gemini新增的製作音樂模組(終於有人挑戰suno了),試了一下做一首30秒的武俠歌曲,完成度也很不錯。gemini給我做的國風武俠電影主題曲07 未來展望:AI發展的新節奏與新挑戰Gemini 3.1 Pro的發佈,不僅是一個產品的升級,更預示著AI行業發展的新節奏。技術迭代的加速度。".1"版本號的出現,意味著技術進步的顆粒度更加精細,迭代頻率更加密集。這要求整個行業建立更加敏捷的研發體系、更加靈活的部署架構、更加智能的測試方法。應用創新的新機遇。更強大的推理能力,將催生更多創新應用場景。從智能教育輔導到專業諮詢服務,從科學計算輔助到複雜決策支援,AI的應用邊界將持續擴展。人才需求的結構性變化。隨著AI能力的快速進化,對AI人才的需求將從"模型訓練專家"向"應用創新專家"轉變。能夠將AI能力與行業需求深度結合的人才,將成為市場的新寵。倫理治理的緊迫性。更強大的推理能力,也帶來了新的倫理挑戰。如何確保AI系統的決策透明、公平、可控,將成為行業必須面對的重要課題。結語Google的這次".1版本突襲",表面上是技術升級,深層則是行業競爭邏輯的根本性轉變。當AI發展從"整數版本躍進"轉向"小數版本迭代",整個行業的節奏、格局、規則都將被重新定義。推理能力的翻倍提升,不僅僅是技術參數的最佳化,更是AI從"資訊處理工具"向"智能思維夥伴"進化的重要里程碑。在這個AI重新定義一切的時代,能夠率先突破推理瓶頸、建構持續最佳化能力的企業,將掌握下一個階段的發展主動權。真正的競爭才剛剛開始。技術優勢需要轉化為生態優勢,單點突破需要擴展為系統領先。對於全球AI產業而言,Gemini 3.1 Pro的發佈既是挑戰,也是機遇。在這個AI從"炫技"走向"實用"的關鍵轉折點,能夠平衡技術創新與商業落地的企業,將引領行業進入更加成熟、務實的新階段。當矽谷醒來時,會發現AI競爭的規則已經改變。這場始於".1版本號"的技術革命,或許將開啟全球AI發展的新篇章——一個更加注重實用性、可及性和可持續性的新篇章。 (遊戲AI說)
科技
#Gemini
#推理能力
#Google
讚
留言
分享
官方認證
RexAA
2026/02/21
•
新德里這場對話,Sam Altman 把 AI 最難的題說透了
AI 能力在加速,這是共識。但真正的問題是什麼?2026 年 2 月 20 日,OpenAI CEO Sam Altman 在新德里的一場訪談裡,給出了他的答案:四道題。能力到那了?算力夠不夠?工作怎麼變?社會跟得上嗎?他沒給標準答案,但把每道題的難點說清楚了。比如 First Proof 為什麼能做對 7 道研究題,Codex 在印度為什麼增長最快,算力瓶頸到底卡在那,工作到底是被替代還是被重寫。拋開字斟句酌的公關話術,這是一次難得的坦率交底。我們整理了訪談的核心內容:AI 能力到那了?算力天花板在那?工作會怎麼變?治理為什麼最難?第一道題|能力到那了:已經跨入“研究級”門檻關於 AI 的真實能力邊界,Altman 強調,過去這一年,模型絕不只是“變聰明了一點”,而是任務難度完全不同了。過去一年,模型從高中數學跨到了研究級數學;從能解釋程式碼,到能生成可運行的應用;從回答物理概念,到推導物理學的新結果。1、從做題到做研究Altman舉了兩個例子: 在 First Proof 實驗(11位頂尖數學家發起的AI測試)中,模型面對10 個研究級數學問題,成功解出了7個。這7道題都有完整推導過程,靠的是邏輯推演。在理論物理學領域,AI也開始推導新的物理學結果,觸及人類知識的前沿。2、工程師的工作重心在變程式設計領域的變化更直觀。很多開發者現在給Codex一個功能描述,它就能生成初版應用:介面、互動、邏輯都有。印度成了全球使用者增長最快的市場。Altman說,大量年輕開發者跳過了傳統程式設計師必經的底層訓練,直接上手就能做出作品。這在開發者群體快速增長的國家特別明顯。3、AGI 已經很接近主持人問到 AGI還有多遠。 Altman的回答很直接:已經很接近了。他給出了一個很有意思的視角:如果時間倒退回六年前,告訴大家有一個系統能做前沿研究、能寫複雜程序、能勝任各種高難度的知識工作,當時的大多數人一定會驚呼“這就是 AGI”。只不過現在,我們身在其中,逐漸對強大的工具習以為常了。按照目前的速度,到 2028 年底,全球 AI 系統同時處理的工作量,可能會超過全人類的總和。從數學、物理、程式設計這些最難突破的領域看,今天 AI 能完成的,已經包括過去只有高技能人才才能處理的知識工作。看懂了今天 AI 這種驚人的能力躍升,我們才能真正明白,為什麼 Altman 接下來會如此急迫地談論“算力瓶頸”。第二道題|算力夠不夠:遠遠不夠主持人問:未來三到五年,AI 最大的限制是什麼?Altman 毫不猶豫地說:算力。 能不能讓足夠多的人,用上足夠強的 AI?這是當下最現實的問題。1、強模型有,但 GPU 不夠用Altman 透露,團隊在實驗室裡看到的模型能力,比公開版本要強得多。之所以沒有全量發佈,是因為算力成本太高。我們有頂級的模型,卻沒有足夠的 GPU 來支撐它全天候為所有人服務。為瞭解決這個問題,OpenAI 在多條線上同時推進:繼續加深與輝達的合作;支援新興晶片公司做推理端的最佳化;同時推進 OpenAI 自己的自研晶片計畫。外界將此解讀為“多線平行”,但 Altman 給的理由極其簡單:要把更強的 AI 推向更廣泛的人群,算力必須大幅擴張。所有能擴產能的路,都必須走。2、真正的天花板:不是水,而是電針對外界流傳甚廣的“每次呼叫 AI 要消耗 17 加侖水”的說法,Altman 明確予以否認。他表示水的使用量被嚴重誇大了,真正需要關注的是能源。他給出了一個對比:訓練一個高智商的人類同樣極其耗能。你需要投入 20 年的時間,以及這 20 年裡他吃掉的所有食物;甚至,還需要算上過去數千代人在進化中學會躲避掠食者、發展出科學,你才有了今天的智慧。相比之下,當模型訓練完成後,AI 回答一個問題的能源效率,其實已經趕上了人類。但真正的挑戰在於“規模”。 下一代資料中心的耗電量將是驚人的。模型越來越龐大,使用者急劇增加,每次呼叫都需要海量晶片協同工作。未來的算力命脈,將極度依賴核能、風能、太陽能,甚至需要為 AI 專門建造超級能源站。3、未來的需求到底有多大?Altman 反問了一個問題:“你個人希望有多少個 GPU 隨時待命為你工作?”答案從來沒有低於過 1 個。甚至有人開口就要 1000 個。試想一下,如果全球 80 億人每人都需要 1000 個專屬 GPU,那就是 80 兆個。這個規模,短期內根本做不到。這意味著,算力需求的上限遠超我們當下的想像。當 AI 徹底融入每個人的工作流,呼叫量將是現在的數十百倍,算力會像今天的水和電一樣,成為最底層的社會基礎設施。這也是為什麼 Altman 感嘆:“擴充算力,可能是人類歷史上最複雜的合作工程。”靠傳統的人力去搞基建,絕對完不成這個任務。好消息是,未來的 AI 和機器人會反過來幫我們建造這些設施。4、基建搞到太空裡?現在還太早。當被問及是否有建造“太空資料中心”的極端可能性時,Altman 明確表示:在目前的情況下,這個想法非常荒謬。發射成本、GPU 的太空維修、能源的穩定供應…… 這些問題一個都還沒解決,近十年內,軌道資料中心都不可能大規模落地。如果說第一道題是在講 AI “能做什麼”,那麼第二道題的核心就是:“你能不能用得上”。 在這場競賽裡,率先掌握穩定且龐大算力的組織,就能拿走下一輪效率革命的入場券。第三道題|工作怎麼變:性質在變,不會消失在對話中,主持人問到最敏感的問題:AI 會讓多少人失去工作?Altman 說,過去一年他看到的變化是:工作沒有消失,但做事方式完全不同了。1、知識型崗位受衝擊最明顯過去一年,程式設計師群體感受最明顯。Altman拿自己舉了個例子:“我本人就是學軟體工程出身的,但我當年學程式設計的那套方法,現在已經徹底過時了。手工編寫C++程式碼的時代,已經結束了。”軟體工程師還需要,但工作內容變了。以前寫程式碼是從零開始搭結構、寫邏輯、偵錯;現在,大段的初版程式碼都由AI一鍵生成,人做的是結構調整、細節修正、風險檢查、體驗提升。這個變化不只發生在程式設計領域。影視創作也一樣:字節跳動 2 月發佈的Seedance 2.0,能從幾句文字描述直接生成電影級視訊片段,導演賈樟柯用它創作了短片《賈樟柯的舞蹈》。大多數知識工作都類似:AI 生成初稿,人負責方向、質量和判斷。2、新機會在那裡?每次技術革命都會洗牌,但最終總會湧現更多的新崗位,只不過這次的浪潮來得更快、更猛。Altman 總結了三個正在發生的趨勢:“超級個體”崛起: 過去開發一個產品需要設計、前端、後端、營運齊上陣;現在,一個人配上一套 AI 工具鏈,就能打造一家完整的“一人公司(OPC)”。創作門檻大幅降低: 不僅僅是程式設計,視訊剪輯、產品設計、文案寫作,過去需要長年專業訓練的技能,現在幾天就能上手。企業內部分工在變: 純做財務的人可以利用 AI 搭建流程自動化系統;不懂程式碼的營運也能直接生成實用的內部工具。用 Altman 的一句話概括就是:“AI 讓很多專業技能變簡單了:以前要專門學,現在會用工具就夠。”3、什麼能力變得更重要?與 AI 深度協作的能力: 會提出好問題(Prompt),會審查生成結果,會組合各種 AI 工具。你要把 AI 當作一個需要磨合的長期合夥人。極致的適應力: 技術迭代在瘋狂加速,過去十年的跨度現在一年就能跑完。能不能在劇變中迅速找到自己的新生態位,是生死攸關的能力。對“人”的深刻理解: AI 再強大,也不知道“什麼樣的設計能直擊人心”、“什麼樣的功能最懂人性的軟肋”。這是人類獨有的嗅覺。此外,Altman 強調了“情感連接”的不可替代性。比如圖像生成 AI 剛出來時,很多人哀嘆插畫師完了。對於批次生產的商業設計(比如生日賀卡)確實如此;但在純藝術領域,AI 生成的畫作價格很低,而人類藝術家創作的作品價格依然在漲。因為人們在乎的是作品背後的那個人。同樣,他提到最近去醫院的經歷,他在意的是護士的細心照料與情感安撫。如果換成一個冷冰冰的機器人,再聰明、再精準,他也會感到排斥。有些工作的核心價值,建立在人與人的連接之上。4、教育方式也在調整既然工作性質變了,教育體系就必須隨之徹底重構。Altman 說,AI 不會讓孩子變懶,關鍵是教學方式能不能跟上工具變化。他回憶起自己上學時,Google剛剛問世。中學老師覺得:如果能直接在Google上查,為什麼還要背歷史日期?他的回答是:死記硬背本來就是浪費時間。幾年後,老師們逐漸接受了,教育系統也在演進。新工具帶來的過程都是這樣:能力提升,要求也提升,我們開始教人們更深入地思考、創造更多。如果學生一直被要求“背內容”、“做重複練習”,自然會被 AI 替代。但如果強調思考方式、項目能力、如何用工具解決問題,AI 反而會讓學習更高效。教育的重點,也將會從“會不會”轉向“怎麼用”。未來的每個人競爭力在於誰能更快把 AI 融入日常工作,讓自己從重複勞動中解放出來,把時間用在更高價值的部分。第四道題|社會跟得上嗎:這是最難的前三道題講了能力、算力、工作。最難的題是:社會跟得上嗎?模型訓練速度在加快,能力在跳躍,可能一年就跨越多代。但社會結構的變化,職業體系、企業流程、法律框架、公共認知,不可能同步跟進。Altman 說:能力提升容易,學會怎麼用才難。1、治理的核心:給社會留出適應時間面對外界對 AI 失控的恐慌,Altman 坦言,他最擔心的是大眾對“治理”的誤解。很多人把監管等同於“阻擋技術前進”,卻忽略了監管的真正目的:是幫助社會打好地基,去安全地擁抱這種前所未有的新能力。他給出了破局的三個關鍵點:逐步開放新功能。新功能上線,使用者學習,行業適應,風險暴露,再調整。這就是“迭代部署”的意義:給社會留出適應時間,不是一次性放開。讓更多人用得起最強工具。如果只有少數人用得起,創新、教育、創業都會受限。普惠既降低風險,也擴大機會。真正的風險來自不會用。模型不懂人類價值,但人懂。問題出在不知道怎麼正確使用,不具備判斷能力,用老辦法應對新工具。2、治理靠分散智慧,各國在探索現在,各個國家正在嘗試不同的監管方法。Altman 認為這是好事:接下來幾年,我們會看到很多不同的嘗試,觀察那些有效、那些無效。世界會傾向於更有效的方法。他尤其強調,當 AI 滲透到千行百業,單靠任何一家科技巨頭,都不可能搞懂所有領域的細節風險。Altman 說:“好的辦法是讓各行各業的人都來討論,而不是只靠科技公司制定規則。”各行各業參與能減少風險,但不能消除不確定性。面對這樣強大的技術,Altman 說,最重要的是保持謙遜。我們最好的猜測也可能是錯的,AI 的發展已經帶來了很多意外,未來還會有更多。結語|說透了什麼這場新德里的訪談,Altman 講了四道題:能力到那了:已經能做研究級工作算力夠不夠:遠遠不夠工作怎麼變:性質在變,不會消失社會跟得上嗎:這是最難的他沒給答案,但把每道題的核心矛盾說清楚了。能力在跨越,算力在追趕,工作在重塑,社會在適應。誰能更快把 AI 融入日常工作,誰就能在這輪變化中佔據主動。 (AI深度研究員)
科技
#Altman
#AI 能力
#算力
讚
留言
分享